Microsoft: MAI-Voice-2
MAI-Voice-2 یک مدل تبدیل متن به گفتار با قابلیت بیانگری بالا از شرکت مایکروسافت است. این مدل برای دستیارهای مکالمهمحور، روایت محتوای رسانهای، ابزارهای دسترسپذیری، آموزش و سایر کاربردهای صوتی با متنهای طولانی مناسب است. قابلیتهای این مدل شامل پشتیبانی از ۱۵ زبان در ۱۸ منطقه جغرافیایی، کنترل دقیق لحن و نحوه بیان، تولید گفتار با صدای گویندگان متعدد و امکان استفاده از نمونههای صوتی کوتاه به عنوان الگو (بدون نیاز به فرآیند تنظیم دقیق یا Fine-tuning) است. اولویت اصلی این مدل، طبیعی بودن و بیانگری گفتار است و نه تولید آن با تأخیر بسیار کم (که در برخی کاربردها حیاتی است).

دسترسی API، ساختهشده برای برنامهنویسها
مشخصات اصلی مدل هوش مصنوعی
| نام مدل | microsoft/mai-voice-2 |
| تاریخ ساخت | ۱۴۰۵/۵/۳۱ |
| سرعت مدل | 3 / 5 |
| Tokenizer | Other |
| Reasoning | غیرفعال |
| هزینه خروجی متن | $0 به ازای هر یک میلیون توکن |
Microsoft: MAI-Voice-2
هر ماه مدلهای هوش مصنوعی متنوعی از شرکتهای مختلف ارائه میشود. ثبت نام، راهاندازی و مدیریت اکانتها و مدیریت مالی مدلهای مختلف کار دشواریست. هوش مصنوعی لیارا، مدلهای برتر دنیا را از طریق یک اکانت و یک کلید دسترسی در اختیار شما قرار میدهد.
مانیتورینگ پیشرفته
تعداد درخواستها، توکنهای مصرفی و هزینههای خود را بهتر مدیریت کنید.
توکن رایگان روزانه
با استفاده از توکنهای رایگان، هزینههای هوشمندسازی نرمافزار خود را کاهش دهید.
مدلهای متنوع
ما به سرعت در حال اضافهکردن مدلهای برتر دنیا هستیم. از OpenAI و DeepSeek گرفته تا Grok و Meta.
معماری مدل
| ورودیها | text |
| خروجی | speech |
| Structured Outputs | غیرفعال |
| Function Calling | غیرفعال |
| Tuning | غیرفعال |
| Streaming | غیرفعال |
پارامترهای قابل تنظیم | max_completion_tokensmax_tokenstemperaturetop_p |
ما سعی میکنیم قابلیتهایی که بهطور مشترک در اکثر مدلها وجود دارد را در قالب OpenAI API پیادهسازی کنیم تا نیازی نباشد برای جابهجایی بین مدلهای مختلف، کدهای خود را تغییر دهید.

